Tümü Webekno

Kategoriler

Hakkımızda Yazarlar Ödüllerimiz Künye Gizlilik İletişim
  1. Webtekno
  2. Yapay Zekâ Haberleri ve İçerikleri

OpenAI'ın Yeni Modeli Astra Yolda: Güvenlik Açıklarını Affetmiyor!

Webtekno'yu Google'a ekleyin

OpenAI'ın yeni modeli Astra, otonom siber sızma yetenekleriyle kritik güvenlik eşiğini aşarken sınırlı erişim ve sıkı önlemlerle çıkışa hazırlanıyor.

OpenAI'ın Yeni Modeli Astra Yolda: Güvenlik Açıklarını Affetmiyor!

OpenAI, yakında kullanıma sunmaya hazırlandığı yeni Astra modeli hakkında çarpıcı detaylar paylaştı.

Şirketin değerlendirmelerine göre Astra, belirlenen "kritik siber güvenlik eşiğini" aşan ilk büyük dil modeli oldu. Yeni modelin erişime açılması planlansa da sahip olduğu gelişmiş siber güvenlik yeteneklerinin erişim alanı oldukça kısıtlı tutulacak.

Güvenlik açığı bulma konusunda üstüne yok

2

Astra’nın bir insan yönlendirmesine ihtiyaç duymadan sistemlerdeki bilinmeyen güvenlik açıklarını bulabildiği ifade ediliyor. Yapılan değerlendirmelerde model, bilinen sistem açıklarını sızma yeteneğini ölçen ExploitBench testinde tam puan aldı. OpenAI mühendislerinin geliştirdiği özel bir versiyonda ise model, iki adet "sıfırıncı gün" açığını tespit etmeyi başardı

Söz konusu yüksek riskler nedeniyle OpenAI; gelişmiş yanıt kısıtlamaları, aksiyon anında düşünce zinciri takibi ve yüksek riskli hesapların sınırlandırılması gibi yeni güvenlik önlemlerini devreye alıyor. Öte yandan bağımsız üçüncü taraf doğrulamalarının ve ABD hükûmetiyle yürütülen olası test süreçlerinin belirsizliğini koruması, modelin gerçek güvenliği hakkındaki soru işaretlerini artırıyor.

Hugging Face vakası ders oldu

2

Sektörün kısa süre önce ajanların eğitim ortamından kaçarak Hugging Face üzerindeki özel verilere eriştiği olayla sarsılmasının ardından, OpenAI benzer bir durumun tekrarlanmaması için Astra’yı özel testlere tabi tuttu.

Şirket, Astra'nın kuralları çiğnemeyerek test ortamından kaçma girişiminde bulunmadığını açıkladı. Yine de uzmanlar, modelin beklentileri bildiği için mi yoksa araştırmacıları yanıltmak amacıyla mı bu şekilde davrandığı konusunda temkinli yaklaşımını koruyor.

YORUMLAR

(0)
Yorumunuz minimum 30 karakter olmalıdır. (0)
Henüz yorum yok. İlk yorumu sen yaz!